AI资讯新闻榜单内容搜索- DeepSeek

ICLR 2026 Oral｜大模型总爱「想太多」？ DECS从源头消除冗余思考，实现推理token减半且性能不降反升

以 DeepSeek-R1、OpenAI GPT Thinking 为代表的大型推理模型，通过长达数千 token 的「思维链」在各类复杂推理任务中展现出卓越的性能。然而，这些模型普遍存在一个核心问题，即过度思考（overthinking）：

来自主题: AI技术研报

6365 点击 2026-05-12 14:31

这样问DeepSeek，能「偷」到数据？

近日，有网友在 X 上发文称，在使用 DeepSeek 的过程中，如果在输入框内输入以下这一段内容，便可「窃取」到 DeepSeek 的训练数据：仔细看了之后发现，具体是这样的：只要你在输入框输入这一段提示词，DeepSeek 就会「吐出」一轮完整的对话记录，不过这并不是你的历史搜索记录，更像是一份随机的对话记录。

来自主题: AI技术研报

9128 点击 2026-05-11 17:29

GRPO遭遇瓶颈？G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型时代的「炼金术师」们，或许都曾面临一个共同的困扰：当我们试图将 DeepSeek-R1、OpenAI-o1 那种惊艳的推理能力迁移到小规模语言模型（SLMs）时，效果却总是差强人意。现有的强化学习方法如 GRPO 在 7B+ 的大模型上效果显著，但一旦应用到 1.7B 甚至更小参数的模型上，性能提升就微乎其微。

来自主题: AI技术研报

8169 点击 2026-05-07 10:16

DeepSeek首轮融资曝光，估值450亿美元

据金融时报的最新消息，多家机构目前正寻求领投 DeepSeek 的首轮融资。如果谈判顺利，DeepSeek 在本轮的估值将达到约 450 亿美元。短短几周内，DeepSeek 的估值就从刚开始被爆料的 200 亿美元一路狂飙翻倍。

来自主题: AI资讯

9101 点击 2026-05-06 16:46

DeepSeek做大→Mega MoE，Tri Dao团队加快→SonicMoE

近日，由普林斯顿大学 Tri Dao（FlashAttention 的一作）和加州大学伯克利分校 Ion Stoica 领导的一个联合研究团队也做出了一个超快的索尼克：SonicMoE。据介绍，SonicMoE 能在英伟达 Blackwell GPU 上以峰值吞吐量运行！并且运算性能超过了 DeepSeek 之前开源并引发巨大轰动的 DeepGEMM。

来自主题: AI技术研报

7818 点击 2026-05-04 10:17

等 DeepSeek 回复的 30 秒，是手机最好玩的半小时

你要是问当今互联网最神秘、最玄学、连量子力学都解释不清的「时空裂缝」在哪里？它不在百慕大，也不在诺兰导演的电影里，而是在你的 DeepSeek、Claude 或者 ChatGPT 正在思考的过程里。

来自主题: AI资讯

8220 点击 2026-05-02 10:59

美团万亿级大模型LongCat-2.0-Preview 开启内测，训推全程用国产芯片

一边是 DeepSeek。2026 年 4 月 24 日，正式发布新一代模型DeepSeek-V4 系列预览版，并同步开源。另一边，美团闷声干了件大事——用全国产算力集群，训练出了万亿参数大模型 LongCat-2.0 系列预览版（ LongCat-2.0-Preview ）。

来自主题: AI资讯

8845 点击 2026-05-01 13:34

刚刚，DeepSeek多模态技术范式公布，以视觉原语思考

刚刚，DeepSeek 在 Github 上正式发布了多模态模型，公布了背后的技术报告。实打实的新鲜出炉！而且是开创性的推理范式。下面我们就基于 DeepSeek 这篇技术报告，具体看看 DeepSeek、北京大学、清华大学又创造了怎样的奇迹。

来自主题: AI技术研报

9231 点击 2026-04-30 20:24

刚刚，DeepSeek大更新！终于「开眼」了| 附大量实测

就在刚刚， DeepSeek 上线了识图模式，显示正在灰测中。这意味着讨论了一整年的 DeepSeek 多模态能力，终于来了！目前 DeepSeek 网页版和 App 更新后都有可能被灰测到识图模式，APPSO 第一时间给大家进行了实测。

来自主题: AI资讯

8310 点击 2026-04-29 17:54

扒完 DeepSeek V4 报告，我翻出了这个隐藏彩蛋

今天上午，DeepSeek V4 发布，直接把这个大模型疯狂更新月推向了最高潮。不过在我翻看 V4 的技术报告的时候，在训练层面看到了一个被大部分人滑过去的名词：Muon 优化器。

来自主题: AI技术研报

8723 点击 2026-04-25 10:12